jina-ocr-v1:在低成本 GPU 上更快解析文档
jina-ocr-v1:在低成本 GPU 上更快解析文档Jina AI 发布端到端文档解析模型 jina-ocr-v1,以 3.4B 总参数/570M 激活参数在 OmniDocBench v1.6 与 olmOCR-Bench 上刷新同级别最佳成绩,并凭借 FastMTP 推测解码与分级密集奖励在低成本 GPU 上实现无损近倍速生成,单页仅输出 1085 个 token 以 2.57 页/秒吞吐领跑 14 款主流系统。
搜索
Jina AI 发布端到端文档解析模型 jina-ocr-v1,以 3.4B 总参数/570M 激活参数在 OmniDocBench v1.6 与 olmOCR-Bench 上刷新同级别最佳成绩,并凭借 FastMTP 推测解码与分级密集奖励在低成本 GPU 上实现无损近倍速生成,单页仅输出 1085 个 token 以 2.57 页/秒吞吐领跑 14 款主流系统。
专注于收集人体运动数据以训练人形机器人的AI机器人初创公司Mecka AI,即将完成由红杉资本领投的新一轮融资,估值约为5亿美元,该公司通过付费让人们佩戴传感器记录日常任务来获取机器人训练所需的真实世界数据。
在具身智能技术路线尚未定型的阶段,基础设施需求正率先收敛,百度智能云以百度百舸AI计算平台为核心,为超过50家具身智能企业提供涵盖模型迭代、数据生产和跨本体部署的全栈AI云支撑,并在《中国具身智能云市场份额报告,2025》中以29.55%份额位居第一。
9 月 18 日,阿里达摩院联合浙江大学医学院附属第一医院等机构研发的通用医疗影像模型 DAMO RADAR 登上《Science》正刊,并正式对外开源。这也是近年来中国 AI 模型罕见登上《Science》正刊。
就在十天前,一部AI短片,在整个AI圈炸了。AI超创DiDi_OK的《网站》,在2026年威尼斯Reply AI Film Festival上拿了双料大奖。76个国家、3100多部作品里杀出来,评委阵容里坐着奥斯卡得主和《狮子王》联合导演。
小布、ColorOS 17 与「AI 硬件」
智谱首席科学家唐杰发布 GLM-5.3-Flash 推理系统优化成果,模型仅用两周在超 10 万颗国产 AI 加速器集群上完成生产部署,端到端吞吐提升 3.2 倍,并由 GLM-5.3 驱动的 Infra Agent 参与瓶颈分析与代码修改,标志着智谱首个 RSI(递归自我改进)早期形态的落地。
你敢信,曾经全力推动 AI 学着说话的人,现在做出了一个「闭嘴」的模型。
想象一下,你正在赶一份 PPT,突然想让 AI 把一张产品图改成海报。
9 月 3 日,OpenAI 正式发布 GPT-6 Astra。在 ARC-AGI-3(一个考验 AI 能否在陌生环境中自主探索、理解规则并规划行动的 Benchmark),Astra 拿下 99.9%,并在 96% 的关卡中达到或超过人类的行动效率基准。